MP
MarkTechPost • 19일 전
IMP 7
메타 FAIR, GPU 낭비 줄이는 AI 연구 선호 모델(RPM) 공개
메타 FAIR이 옥스퍼드대·UCL과 함께 AI 연구 선호 모델(RPM)을 발표했습니다. RPM은 고정된 LLM 심판 역할을 하여 아직 실행하지 않은 15개 실험 후보를 평가·순위화하고 그중 하나만 실제로 실행합니다. AIRS-Bench에서 평균 정규화 점수가 0.684에서 0.729로 상승했고, 기존 24시간 걸리던 결과가 약 15시간 만에 도달해 비용 효율적인 자동 AI 연구에 중요한 진전입니다.
메타 FAIR 선호 모델 AI 연구 에이전트